DeepSeek V4正式版测试视频曝光,或于下周一发布,承接Kimi K3热度。实测性能对标Claude Opus4.8,核心指标惊艳,引发行业关注。
马斯克宣布Grok4.5模型在SpaceX与特斯拉内部启动Beta测试,基于1.5万亿参数V9模型,训练中融入Cursor编程数据,性能已接近或超越Claude Opus,强化学习仍在优化中。
火山引擎Force大会上,豆包大模型发布旗舰版本Doubao-Seed-2.1 Pro。基准测试显示其性能已比肩GPT-5.5、Claude Opus 4.7与Gemini 3.1 Pro等国际顶尖模型,标志着国产大模型在核心性能和工程化应用上取得关键突破,非仅参数堆叠。
美国大模型公司Anthropic发布Claude Opus 4.8,虽在多项榜单表现优异,但被曝出认知混乱问题。网友通过API测试发现,该模型在询问身份时,会错误自称是阿里巴巴的“千问(Qwen)”或“DeepSeek”等中国开源大模型,引发关注。